大模型开始卷「越狱」了
大模型开始卷「越狱」了最近,「越狱」这个有点古典的词,又在 AI 圈火了起来。7 月,OpenAI 在进行模型测试时,GPT-5.6 Sol 和另一款待发布的模型,攻击了第三方开源平台 Hugging Face。先是 Hugging Face 自己发布了报告,提到相关服务遭到了完全由 AI Agent 组织的大规模网络攻击;随后 OpenAI 出来认领,「我就是那个发起攻击的 AI 模型。」
搜索
最近,「越狱」这个有点古典的词,又在 AI 圈火了起来。7 月,OpenAI 在进行模型测试时,GPT-5.6 Sol 和另一款待发布的模型,攻击了第三方开源平台 Hugging Face。先是 Hugging Face 自己发布了报告,提到相关服务遭到了完全由 AI Agent 组织的大规模网络攻击;随后 OpenAI 出来认领,「我就是那个发起攻击的 AI 模型。」
就在刚刚,Meta Superintelligence Labs 正式发布 Muse Glimmer,一个 300 亿参数的开源权重 Agent 模型,并直接挂上相当宽松的 Apache 2.0 许可证。Muse Spark 1.2 的权重也会开放
Runta 是 Agent Infra 领域的硅谷明星创业公司,刚完成由 a16z 投资的 2000 万美元 Seed 轮;Jeff Dean、李飞飞等也以个人天使身份参与投资。在创立 Runta 之前,冠兰在云计算与基础设施领域深耕十余年:曾任 Cloudflare Edge 边缘云核心技术负责人,后在作为早期核心成员加入 Kong ,担任工程总监,负责云原生网关和 AI 网关的研发。
一场开发者封号风波,最后演变成了 OpenAI 和 Anthropic 两位 Coding Agent 负责人之间的一场大型公开“互怼”。
过去两年,self-reflection、self-correction、self-play、agentic RL、skill learning、test-time adaptation、open-ended evolution、self-evolving agent等概念不断涌现。
MiniMax 在发布说明里直接用了两个词:Rebuilt on Pi Agent,基于开源 Pi Agent 框架重构;宣传图上写得更干脆,Rebuilt from the Core,从核心重建。对 Node.js 开发者来说,这件事比又一款 AI 编程工具上线更有意思。
7月22日,美国某研究审查公司用AI Agent对ICML 2026全部168篇口头报告论文进行了系统性的结果复现审计。168篇论文中有92篇拥有至少5条可供验证的结论性声明。最终的结果是:AI Agent能够成功复现超过四成结论的,只有34篇;而能复现八成以上结论的,仅有8篇。
Cloudflare 用 12 周从零写了一个浏览器。Rust 编写,跑在自家的 Workers 边缘网络上,内存占用最多比 Chromium 省 7 倍,专给 AI agent 用,beta 期免费。名字叫 Kitesurf。官博和推文里反复念叨同一句话,Chromium 太沉了,没法给每个 agent 都发一个。
2026 年 1 月,Floatboat 客户端把文件管理器、编辑器和浏览器直接做成 Agent 的运行环境,开创了 Agent 桌面工作台这一形态;4 月,FloatIM 把人与 Agent、Agent 与 Agent 接成一张办公网络,任务可以跨人、跨 Agent 交接而上下文不断;5 月,FloatSchedule 让 Agent 不必等人下指令,按日程自己开工。
这个框架名叫 Prime Agent,由 Prime Intellect 发布。官方对它的定义是:一个面向编程、研究和长时间自主任务的「自我改进 RLM harness」。RLM 是 MIT 博士生 Alex Zhang 等人去年 10 月发布的一项工作(参见《递归语言模型登场!MIT华人新作爆火,扩展模型上下文便宜又简单》)